Umešao se u nerešeno ubistvo! Četbot otišao na sajt policije, otvorio formular za građane i šokirao
Dodajte Kurir u vaš Google izbor- AI kompanije Anthropic poslala je lažnu dojavu o ubistvu preko formulara sajta policije u Filadelfiji tokom internog testiranja.
- Model Claude Haiku 4.5 trebalo je da simulira interakciju sa sajtom, ali je stvarno poslao poruku kroz javni obrazac.
- Policija je prijavu označila kao spam, pa nije stigla do istražitelja, dok je Anthropic kasnije ograničio pristup internetu za AI agente.
Prijava je poslata preko sajta PhillyUnsolvedMurders.com, koji služi za prikupljanje informacija o nerešenim ubistvima. Policijski sistem označio je poruku kao neželjeni sadržaj, pa ona nije prosleđena istražiteljima.
Prema informacijama koje je objavila kompanija, model Claude tokom zadatka trebalo je da napravi primer interakcije sa internet stranicom, ali je umesto toga zaista poslao sadržaj kroz formular za prijavu.
Policijska uprava Filadelfije kritikovala je činjenicu da je o događaju obaveštena tek nakon više od dva meseca, dok je Anthropic naveo da je nakon otkrivanja problema ograničio pristup internetu za AI agente tokom internih testiranja i počeo da preispituje bezbednosne mere koje sprečavaju ovakve radnje.
Model koji je učestvovao u incidentu zove se Claude Haiku 4.5. Prema izveštaju kompanije Anthropic, sistem je tokom internog testiranja dobijao zadatke koji su podrazumevali interakciju sa nasumično izabranim internet stranicama. Kada je naišao na sajt policije Filadelfije, otvorio je formular namenjen građanima i poslao izmišljenu informaciju o nerešenom ubistvu.
Uputstva za testiranje zabranjivala su modelu da se prijavljuje na naloge, pravi nove korisničke naloge, unosi lične podatke, obavlja kupovine ili preduzima određene štetne radnje. Međutim, slanje internet formulara nije bilo izričito zabranjeno. Model je zato mogao da izvrši radnju koja nije bila predviđena, iako je zadatak bio zamišljen kao testiranje rada na različitim sajtovima.
Zašto prijava nije stigla do istražitelja?
Poruka je poslata preko javno dostupnog formulara, a ne upadom u policijsku mrežu. Policijski sistem automatski ju je prepoznao kao neželjeni sadržaj i zadržao u folderu za spam. Srećom, zbog toga prijava nije prosleđena Real-Time Crime Centeru, tj. centru koji prima i procenjuje informacije relevantne za policijske istrage.
Policija je navela da nije pronašla dokaze o neovlašćenom pristupu svojim sistemima niti o kompromitovanju podataka. Ipak, lažne dojave mogu da opterete službe i skrenu pažnju sa stvarnih informacija, posebno kada je reč o nerešenim zločinima. U ovom slučaju, automatski filter sprečio je da izmišljena poruka stigne do istražitelja koji bi morali da procene njenu relevantnost.
Kompanija je za incident saznala tek u septembru
Prema podacima koje je policija objavila, lažna prijava poslata je 18. jula u 23.27 časova po lokalnom vremenu. Anthropic je tek 28. septembra utvrdio da je tokom testiranja došlo do slanja poruke preko policijskog formulara. Nakon otkrivanja problema, kompanija je prekinula automatizovani proces testiranja koji je doveo do incidenta.
Policija Filadelfije obaveštena je 7. oktobra, a predstavnici kompanije i policije sastali su se narednog dana. Policijska uprava javno je kritikovala dvomesečno kašnjenje u otkrivanju i prijavljivanju događaja. Anthropic je, prema dostupnim informacijama, uveo dodatnu proveru za buduće testove kako bi smanjio mogućnost da automatizovani sistem neplanirano šalje sadržaj stvarnim internet servisima.
AI agenti mogu da rade više od pisanja odgovora
Inače, za razliku od običnog četbota koji samo sastavlja tekst, AI agent može da koristi digitalne alate i izvršava niz koraka na internetu. U zavisnosti od pristupa koji mu je omogućen, može da otvara stranice, prikuplja informacije, popunjava formulare i šalje podatke. Takve mogućnosti mogu da olakšaju svakodnevne poslove, ali zahtevaju precizna ograničenja kako bi se sprečilo da agent obavi radnju koju korisnik ili programer nije nameravao.
Slučaj iz Filadelfije nije bio jedini incident koji je Anthropic prijavio. U izveštaju objavljenom u oktobru 2026. kompanija je opisala i druge situacije u kojima su njeni modeli tokom testiranja preduzimali neželjene radnje na internet stranicama, uključujući državne servise.
Zabranjeno preuzimanje dela ili čitavog teksta i/ili foto/videa, bez navođenja i linkovanja izvora i autora, a u skladu sa odredbama WMG uslova korišćenja i Zakonom o javnom informisanju i medijima.